model.embed_tokens.weight_quantizer TensorQuantizer(disabled) model.embed_tokens.input_quantizer HardDisabledTensorQuantizer(disabled) model.embed_tokens.output_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.0.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.0.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.0.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.0.mlp.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.0.mlp.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.0.mlp.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.0.mlp.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.0.mlp.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.0.mlp.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.0.mlp.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.0.mlp.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.0.mlp.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.1.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.1.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.1.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.1.mlp.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.1.mlp.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.1.mlp.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.1.mlp.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.1.mlp.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.1.mlp.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.1.mlp.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.1.mlp.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.1.mlp.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.2.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.2.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.2.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.2.mlp.experts.gate_up_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_input_quantizer TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.2.mlp.experts.down_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.2.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.3.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.3.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.3.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.3.mlp.experts.gate_up_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_input_quantizer TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.3.mlp.experts.down_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.3.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.4.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.4.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.4.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.4.mlp.experts.gate_up_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_input_quantizer TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.4.mlp.experts.down_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.4.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.5.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.5.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.5.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.5.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.59e+00 calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.92e+01 calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0036, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.5.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.5.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.5.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.5.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.5.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.5.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.5.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.5.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.5.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.6.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.6.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.6.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.6.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.28e+00 calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.20e+01 calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.6.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.6.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.6.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.6.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.6.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.6.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.6.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.6.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.6.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.7.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.7.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.7.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.7.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.00e+00 calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0025, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.02e+01 calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0014, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0000, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.7.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.7.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.7.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.7.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.7.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.7.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.7.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.7.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.7.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.8.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.8.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.8.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.8.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.47e+00 calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.31e+02 calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.8.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.8.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.8.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.8.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.8.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.8.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.8.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.8.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.8.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.9.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.9.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.9.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.9.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.75e+00 calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0036, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.14e+02 calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.9.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.9.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.9.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.9.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.9.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.9.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.9.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.9.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.9.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.10.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.10.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.10.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.10.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.12e+00 calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.28e+02 calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0000, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.10.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.10.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.10.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.10.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.10.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.10.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.10.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.10.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.10.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.11.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.11.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.11.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.11.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.69e+00 calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.60e+02 calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 1.0000](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 1.0000](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.11.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.11.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.11.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.11.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.11.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.11.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.11.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.11.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.11.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.12.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.12.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.12.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.12.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.15e+01 calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.20e+01 calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.12.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.12.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.12.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.12.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.12.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.12.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.12.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.12.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.12.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.13.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.13.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.13.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.13.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.23e+01 calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.00e+02 calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.8125](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.8125](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 1.2500](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 1.2500](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.13.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.13.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.13.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.13.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.13.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.13.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.13.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.13.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.13.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.14.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.14.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.14.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.14.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.07e+01 calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.10e+02 calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.9375](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.9375](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.14.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.14.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.14.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.14.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.14.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.14.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.14.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.14.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.14.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.15.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.15.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.15.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.15.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.22e+01 calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.75e+01 calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.15.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.15.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.15.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.15.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.15.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.15.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.15.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.15.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.15.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.16.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.16.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.16.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.16.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.04e+01 calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0058, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.17e+02 calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.16.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.16.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.16.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.16.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.16.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.16.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.16.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.16.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.16.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.17.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.17.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.17.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.17.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.04e+01 calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.34e+02 calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.17.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.17.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.17.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.17.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.17.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.17.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.17.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.17.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.17.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.18.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.18.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.18.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.18.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.01e+01 calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.10e+02 calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.8750](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.8750](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.18.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.18.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.18.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.18.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.18.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.18.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.18.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.18.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.18.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.19.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.19.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.19.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.19.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.62e+00 calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.05e+01 calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.19.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.19.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.19.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.19.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.19.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.19.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.19.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.19.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.19.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.20.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.20.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.20.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.20.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.56e+00 calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.30e+01 calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.20.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.20.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.20.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.20.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.20.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.20.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.20.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.20.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.20.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.21.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.21.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.21.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.21.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.53e+00 calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0014, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=8.95e+01 calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.21.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.21.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.21.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.21.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.21.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.21.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.21.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.21.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.21.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.22.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.22.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.22.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.22.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.38e+00 calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.2188](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.2188](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.16e+02 calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 1.1250](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 1.1250](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.22.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.22.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.22.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.22.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.22.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.22.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.22.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.22.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.22.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.23.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.23.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.23.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.23.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.94e+00 calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2188](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.56e+02 calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 1.0000](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.9375](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.23.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.23.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.23.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.23.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.23.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.23.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.23.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.23.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.23.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.24.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.24.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.24.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.24.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.14e+01 calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.67e+02 calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.24.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.24.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.24.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.24.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.24.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.24.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.24.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.24.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.24.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.25.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.25.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.25.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.25.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.44e+01 calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0025, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.12e+02 calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2188](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.25.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.25.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.25.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.25.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.25.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.25.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.25.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.25.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.25.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.26.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.26.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.26.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.26.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.32e+01 calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.2188](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.2188](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.28e+02 calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 1.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 1.1250](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.26.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.26.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.26.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.26.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.26.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.26.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.26.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.26.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.26.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.27.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.27.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.27.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.27.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.41e+01 calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2812](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.68e+02 calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4375](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.9375](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.9375](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.4062](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.27.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.27.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.27.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.27.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.27.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.27.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.27.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.27.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.27.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.28.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.28.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.28.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.28.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.12e+01 calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.74e+02 calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.28.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.28.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.28.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.28.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.28.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.28.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.28.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.28.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.28.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.29.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.29.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.29.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.29.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.58e+01 calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.12e+02 calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.29.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.29.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.29.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.29.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.29.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.29.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.29.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.29.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.29.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.30.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.30.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.30.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.30.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.79e+01 calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.2188](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.2031](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0014, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.2812](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.2812](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.20e+03 calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.8750](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.8125](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.8125](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.30.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.30.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.30.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.30.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.30.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.30.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.30.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.30.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.30.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.31.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.31.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.31.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.31.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.80e+01 calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.10e+01 calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.31.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.31.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.31.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.31.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.31.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.31.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.31.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.31.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.31.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.32.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.32.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.32.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.32.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=2.15e+01 calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0053, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=2.60e+02 calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.32.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.32.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.32.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.32.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.32.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.32.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.32.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.32.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.32.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.33.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.33.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.33.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.33.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=2.31e+01 calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.20e+01 calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.33.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.33.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.33.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.33.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.33.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.33.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.33.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.33.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.33.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.34.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.34.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.34.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.34.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=2.25e+01 calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1875](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1875](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.76e+02 calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3750](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.34.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.34.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.34.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.34.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.34.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.34.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.34.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.34.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.34.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.35.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.35.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.35.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.35.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=2.01e+01 calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.38e+01 calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.35.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.35.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.35.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.35.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.35.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.35.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.35.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.35.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.35.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.36.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.36.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.36.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.36.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=2.39e+01 calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.72e+02 calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0025, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.36.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.36.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.36.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.36.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.36.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.36.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.36.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.36.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.36.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.37.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.37.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.37.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.37.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.19e+01 calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.75e+01 calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.37.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.37.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.37.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.37.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.37.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.37.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.37.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.37.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.37.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.38.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.38.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.38.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.38.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.25e+01 calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=2.42e+02 calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.38.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.38.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.38.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.38.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.38.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.38.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.38.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.38.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.38.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.39.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.39.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.39.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.39.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.42e+01 calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.08e+02 calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.39.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.39.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.39.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.39.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.39.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.39.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.39.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.39.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.39.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.40.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.40.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.40.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.40.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.38e+01 calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.72e+01 calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.40.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.40.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.40.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.40.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.40.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.40.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.40.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.40.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.40.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.41.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.41.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.41.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.41.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.32e+01 calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.90e+01 calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.41.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.41.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.41.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.41.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.41.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.41.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.41.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.41.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.41.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.42.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.42.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.42.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.42.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.42e+01 calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0053, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.78e+02 calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.42.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.42.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.42.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.42.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.42.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.42.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.42.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.42.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.42.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.43.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.43.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.43.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.43.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.70e+01 calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.45e+01 calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.43.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.43.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.43.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.43.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.43.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.43.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.43.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.43.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.43.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.44.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.44.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.44.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.44.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.95e+01 calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.70e+01 calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.44.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.44.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.44.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.44.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.44.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.44.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.44.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.44.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.44.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.45.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.45.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.45.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.45.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.60e+01 calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.21e+02 calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.45.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.45.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.45.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.45.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.45.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.45.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.45.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.45.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.45.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.46.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.46.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.46.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.46.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.48e+01 calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0053, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.08e+02 calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.46.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.46.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.46.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.46.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.46.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.46.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.46.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.46.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.46.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.47.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.47.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.47.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.47.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.42e+01 calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.05e+02 calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.47.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.47.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.47.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.47.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.47.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.47.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.47.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.47.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.47.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.48.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.48.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.48.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.48.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.80e+01 calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.3125](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.3125](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.10e+02 calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.48.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.48.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.48.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.48.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.48.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.48.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.48.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.48.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.48.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.49.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.49.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.49.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.49.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.15e+01 calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.68e+01 calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.49.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.49.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.49.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.49.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.49.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.49.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.49.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.49.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.49.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.50.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.50.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.50.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.50.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.25e+01 calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.38e+01 calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.50.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.50.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.50.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.50.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.50.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.50.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.50.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.50.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.50.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.51.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.51.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.51.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.51.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.58e+01 calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.10e+01 calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.51.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.51.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.51.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.51.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.51.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.51.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.51.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.51.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.51.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.52.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.52.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.52.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.52.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.98e+01 calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.3125](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.2812](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=3.08e+02 calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.52.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.52.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.52.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.52.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.52.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.52.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.52.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.52.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.52.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.53.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.53.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.53.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.53.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.32e+01 calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.01e+02 calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.53.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.53.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.53.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.53.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.53.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.53.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.53.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.53.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.53.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.54.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.54.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.54.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.54.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.60e+01 calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.44e+02 calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.54.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.54.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.54.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.54.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.54.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.54.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.54.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.54.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.54.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.55.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.55.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.55.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.55.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.50e+01 calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.04e+02 calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.55.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.55.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.55.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.55.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.55.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.55.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.55.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.55.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.55.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.56.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.56.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.56.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.56.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.55e+01 calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=9.15e+01 calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.56.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.56.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.56.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.56.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.56.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.56.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.56.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.56.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.56.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.57.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.57.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.57.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.57.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.05e+01 calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.90e+01 calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.57.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.57.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.57.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.57.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.57.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.57.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.57.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.57.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.57.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.58.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.58.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.58.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.58.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.82e+01 calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.78e+01 calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.58.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.58.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.58.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.58.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.58.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.58.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.58.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.58.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.58.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.59.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.59.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.59.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.59.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.00e+01 calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.40e+01 calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.59.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.59.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.59.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.59.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.59.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.59.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.59.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.59.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.59.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.60.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.60.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.60.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.60.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.20e+01 calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=8.80e+01 calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.60.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.60.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.60.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.60.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.60.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.60.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.60.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.60.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.60.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.61.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.61.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.61.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.61.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.98e+01 calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=1.70e+02 calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0058, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.61.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.61.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.61.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.61.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.61.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.61.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.61.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.61.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.61.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.62.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.62.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.62.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.62.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.05e+01 calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.62.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.62.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.62.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.62.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.62.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.62.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.62.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.62.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.62.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.63.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.63.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.63.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.63.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.02e+01 calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.63.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.63.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.63.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.63.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.63.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.63.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.63.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.63.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.63.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.64.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.64.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.64.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.64.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.72e+01 calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.64.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.64.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.64.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.64.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.64.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.64.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.64.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.64.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.64.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.65.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.65.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.65.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.65.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.40e+01 calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.4688](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.65.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.65.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.65.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.65.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.65.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.65.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.65.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.65.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.65.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.66.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.66.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.66.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.66.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.98e+01 calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0019, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.66.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.66.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.66.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.66.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.66.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.66.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.66.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.66.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.66.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.67.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.67.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.67.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.67.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=5.82e+01 calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.67.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.67.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.67.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.67.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.67.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.67.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.67.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.67.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.67.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.68.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.68.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.68.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.68.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=6.22e+01 calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.68.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.68.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.68.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.68.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.68.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.68.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.68.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.68.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.68.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.69.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.69.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.69.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.69.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.25e+01 calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.5625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.69.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.69.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.69.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.69.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.69.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.69.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.69.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.69.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.69.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.70.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.70.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.70.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.70.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.50e+01 calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.2031](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.2031](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.7500](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.70.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.70.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.70.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.70.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.70.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.70.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.70.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.70.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.70.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.71.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.71.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.71.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.71.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.55e+01 calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0586](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0036, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.71.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.71.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.71.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.71.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.71.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.71.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.71.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.71.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.71.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.72.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.72.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.72.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.72.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.80e+01 calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0018, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2500](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3438](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.72.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.72.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.72.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.72.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.72.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.72.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.72.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.72.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.72.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.73.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.73.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.73.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.73.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=8.20e+01 calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.1094](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1406](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0012, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2031](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.2812](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.6875](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.73.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.73.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.73.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.73.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.73.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.73.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.73.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.73.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.73.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.74.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.74.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.74.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.74.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=7.85e+01 calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0003, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.4062](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.4688](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1562](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0004, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1719](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0011, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1250](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0859](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0005, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.1016](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.1172](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0938](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0008, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0006, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0625](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0001, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0007, 0.0781](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0002, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.gate_up_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0010, 0.0703](1572864) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_input_quantizer TensorQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'dynamic', 'scale_bits': (4, 3)}, amax=4.90e+01 calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.0 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.1 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.2 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.3 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.4 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.5 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.6 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.7 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.8 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.9 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.10 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.11 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.12 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.13 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.14 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.15 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.16 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.17 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.18 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.19 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.20 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.21 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.22 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.23 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.24 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.25 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.26 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.27 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.28 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.29 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.30 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.31 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.32 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.33 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.34 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.35 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.36 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.37 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.38 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.39 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.40 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.41 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.42 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.43 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.44 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.45 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.46 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.47 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.48 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.49 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.50 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.51 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.52 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.53 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.54 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.55 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.56 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.57 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1875](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.58 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.59 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.60 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.61 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.62 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.63 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.64 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.65 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.66 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.67 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0024, 0.6250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.68 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.69 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.70 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.71 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.72 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.73 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.74 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.75 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.76 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.77 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.78 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.79 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.80 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.81 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.82 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.83 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.84 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.85 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.86 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.87 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0032, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.88 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.89 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.90 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.91 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.92 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.93 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.94 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.95 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.96 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.97 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.98 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0009, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.99 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0015, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.100 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.101 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.102 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.103 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.104 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.105 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.106 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.107 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1719](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.108 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.109 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.110 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.111 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.112 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.113 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.114 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.115 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.116 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.117 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.118 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.119 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.120 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.121 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.122 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.123 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.124 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.125 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.5000](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.126 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.127 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.128 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.129 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.130 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.131 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.132 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.133 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.134 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.135 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.136 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.137 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.138 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.139 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.140 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.141 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.142 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.143 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.144 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.145 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.146 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.147 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0017, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.148 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.149 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.2344](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.150 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0022, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.151 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.152 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.153 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.154 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.155 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.3125](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.156 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.157 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.158 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.159 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1562](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.160 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.161 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.162 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.163 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.164 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.165 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.166 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.167 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.168 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.169 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.170 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.171 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.172 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.173 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.174 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.175 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.176 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.177 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.178 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.179 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.180 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.181 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.182 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.183 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.184 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.185 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.186 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.187 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.188 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.189 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.190 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.191 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.192 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.193 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.194 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.195 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.196 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.197 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.198 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0013, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.199 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.200 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.201 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.202 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.203 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.204 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1094](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.205 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.206 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.207 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.208 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.209 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.210 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.211 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0027, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.212 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.213 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.214 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0034, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.215 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0029, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.216 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0016, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.217 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0020, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.218 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.219 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.220 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.221 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.222 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.1016](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.223 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.224 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0078, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.225 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.226 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.227 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.228 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.229 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.230 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.231 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.232 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.233 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0938](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.234 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0044, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.235 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0037, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.236 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.237 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0039, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.238 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.239 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1250](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.240 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.241 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0073, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.242 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.243 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0625](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.244 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.245 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0049, 0.0703](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.246 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0859](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.247 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.248 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.249 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.250 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.251 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0063, 0.1172](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.252 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.253 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0059, 0.0781](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.254 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0054, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.experts.down_proj_weight_quantizers.255 StaticBlockScaleQuantizer((2, 1) bit fake block_sizes={-1: 16, 'type': 'static', 'scale_bits': (4, 3)}, amax=[0.0068, 0.1406](786432) calibrator=MaxCalibrator quant) model.layers.74.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.74.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.74.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.74.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.74.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.74.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.74.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.74.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.74.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.75.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.75.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.75.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.75.mlp.experts.gate_up_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_input_quantizer TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.75.mlp.experts.down_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.75.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.76.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.76.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.76.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.76.mlp.experts.gate_up_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_input_quantizer TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.76.mlp.experts.down_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.76.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.q_proj.input_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.q_proj.output_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.q_proj.weight_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.k_proj.input_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.k_proj.output_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.k_proj.weight_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.v_proj.input_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.v_proj.output_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.v_proj.weight_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.o_proj.input_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.o_proj.output_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.o_proj.weight_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.q_bmm_quantizer TensorQuantizer(disabled) model.layers.77.self_attn.k_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.77.self_attn.v_bmm_quantizer TensorQuantizer((4, 3) bit fake per-tensor amax=4.48e+02(const) calibrator=MaxCalibrator quant) model.layers.77.self_attn.p_bmm_quantizer TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_input_quantizer TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.77.mlp.experts.gate_up_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_input_quantizer TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.0 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.1 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.2 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.3 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.4 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.5 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.6 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.7 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.8 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.9 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.10 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.11 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.12 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.13 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.14 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.15 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.16 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.17 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.18 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.19 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.20 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.21 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.22 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.23 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.24 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.25 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.26 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.27 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.28 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.29 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.30 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.31 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.32 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.33 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.34 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.35 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.36 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.37 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.38 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.39 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.40 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.41 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.42 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.43 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.44 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.45 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.46 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.47 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.48 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.49 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.50 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.51 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.52 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.53 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.54 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.55 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.56 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.57 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.58 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.59 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.60 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.61 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.62 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.63 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.64 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.65 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.66 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.67 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.68 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.69 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.70 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.71 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.72 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.73 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.74 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.75 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.76 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.77 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.78 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.79 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.80 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.81 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.82 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.83 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.84 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.85 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.86 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.87 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.88 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.89 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.90 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.91 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.92 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.93 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.94 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.95 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.96 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.97 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.98 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.99 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.100 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.101 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.102 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.103 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.104 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.105 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.106 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.107 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.108 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.109 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.110 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.111 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.112 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.113 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.114 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.115 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.116 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.117 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.118 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.119 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.120 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.121 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.122 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.123 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.124 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.125 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.126 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.127 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.128 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.129 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.130 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.131 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.132 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.133 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.134 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.135 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.136 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.137 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.138 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.139 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.140 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.141 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.142 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.143 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.144 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.145 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.146 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.147 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.148 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.149 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.150 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.151 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.152 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.153 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.154 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.155 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.156 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.157 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.158 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.159 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.160 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.161 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.162 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.163 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.164 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.165 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.166 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.167 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.168 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.169 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.170 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.171 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.172 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.173 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.174 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.175 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.176 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.177 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.178 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.179 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.180 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.181 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.182 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.183 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.184 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.185 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.186 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.187 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.188 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.189 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.190 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.191 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.192 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.193 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.194 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.195 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.196 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.197 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.198 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.199 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.200 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.201 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.202 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.203 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.204 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.205 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.206 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.207 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.208 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.209 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.210 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.211 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.212 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.213 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.214 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.215 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.216 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.217 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.218 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.219 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.220 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.221 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.222 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.223 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.224 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.225 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.226 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.227 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.228 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.229 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.230 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.231 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.232 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.233 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.234 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.235 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.236 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.237 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.238 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.239 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.240 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.241 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.242 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.243 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.244 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.245 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.246 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.247 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.248 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.249 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.250 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.251 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.252 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.253 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.254 TensorQuantizer(disabled) model.layers.77.mlp.experts.down_proj_weight_quantizers.255 TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.gate_proj.input_quantizer TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.gate_proj.output_quantizer TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.gate_proj.weight_quantizer TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.up_proj.input_quantizer TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.up_proj.output_quantizer TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.up_proj.weight_quantizer TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.down_proj.input_quantizer TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.down_proj.output_quantizer TensorQuantizer(disabled) model.layers.77.mlp.shared_experts.down_proj.weight_quantizer TensorQuantizer(disabled) lm_head.input_quantizer TensorQuantizer(disabled) lm_head.output_quantizer TensorQuantizer(disabled) lm_head.weight_quantizer TensorQuantizer(disabled) 41020 TensorQuantizers found in model